#Douglas Lenat
RexAA
官方認證
RexAA
2026/09/20
•已編輯

這是一篇把"RSI"講明白的科普級綜述!

如果你是第一次聽說 RSI,這篇文章可以當作一份入門指南。我們會帶大家把 RSI 從 0 理一遍,從最早嘗試自我改進的 AI 講起,聊到今天能改程式碼、造訓練資料、參與模型研發的 Agent,看看 AI 如何一步步學著改進自己的。 2026 年 7 月,OpenAI 發佈 GPT-5.6。它的成績單裡,第一次出現了一門有些反常的新科目:AI 能不能參與改進 AI 本身。 OpenAI 把這項能力列為自我改進(Self-improvement)。GPT-5.6 Sol 得到 57.9%,GPT-5.5 是 41.7%,兩代模型相差 16.2 個百分點。它考的不是模型又會做多少道常規題,而是它能不能走進 AI 研發現場:排查研究系統、最佳化 GPU 核心程序(GPU kernel)和訓練配方、運行機器學習實驗,甚至幫助改進另一個模型。 這不是一條孤立的新聞。同一個夏天,OpenAI 開始把智能體(Agent)稱為“自動化研究實習生”。快手 AgentX 已經讓智能體參與提出方案、寫程式碼和線上新舊版本對照(A/B 測試)。Google 表示,長期運行的智能體循環參與了下一版模型的精煉。Motus2 則把預測、評估和策略更新帶進了真實機器人。
這是一篇把"RSI"講明白的科普級綜述!
科技#RSI#遞迴增益#遞迴自我改進